Stepfun
-
输入tokens/百万
输出tokens/百万
上下文长度
Baidu
zelk12
这是一个使用mergekit工具合并的预训练语言模型,采用DARE TIES方法融合了多个Gemma3-12B变体模型。
grimjim
MagTie-v1-12B是一个基于DARE TIES算法合并的12B参数语言模型,融合了多个预训练模型的优势
本项目使用mergekit和DARE TIES方法合并了soob3123/amoral-gemma3-12B-v2和IlyaGusev/saiga_gemma3_12b两个模型,旨在提供更强大的语言处理能力。
Tarek07
这是一个基于LLaMa-70B架构的多模型融合实验项目,采用DARE TIES融合方法,结合了6个不同版本的MO-MODEL模型。
ReadyArt
这是一个基于DARE TIES方法合并的12B参数语言模型,融合了多个预训练模型,旨在提供强大的文本生成能力。
这是一个基于Gemma-2-9B系列模型通过DARE TIES方法融合的9B参数规模语言模型,融合了多个优化版本的Gemma模型。
这是一个使用mergekit和DARE TIES方法合并的预训练语言模型,基于多个Gemma-2-9B变体模型融合而成。
这是一个基于Gemma-2-9B系列模型的融合模型,采用DARE TIES方法融合了多个Gemma变体,旨在提升文本生成能力。
这是一个基于Gemma-2-9B系列模型通过DARE TIES方法合并的多模型融合版本,整合了多个Gemma变体的优势。
TareksTesting
使用 DARE TIES 方法合并的预训练语言模型,基于 L-BASE-V1 融合多个 MERGE 模型
darkc0de
这是一个基于 Mistral-Small-24B-Instruct-2501 的融合模型,采用了 DARE TIES 融合方法,整合了多个 24B 参数规模的模型。
DavidAU
一个用于创意、头脑风暴、角色扮演、长篇故事、场景及虚构内容生成的模型,以独特方式融合多个模型,生成极具创意且不可预测的文本内容。
rmihaylov
基于Meta-Llama-3-8B和Meta-Llama-3-8B-Instruct模型,采用DARE TIES合并方法创建的预训练语言模型
BioMistral
BioMistral-MedMNX 是一个通过融合多个预训练模型而创建的生物医学领域专用语言模型,采用 DARE 和 TIES 融合方法优化性能。
jambroz
这是一个使用mergekit工具通过DARE TIES方法合并的7B参数规模语言模型,融合了多个高性能开源模型。
Natkituwu
Erosumika-7B-v3是一个7.1bpw exl2量化的语言模型,适合在8GB显存的GPU上运行16k上下文。它是通过DARE TIES方法融合多个模型而成,主要用于娱乐性质的虚构写作。
sophosympatheia
Midnight Rose是通过DARE TIES方法融合多个70B参数模型而成的创意写作专用大语言模型,在角色扮演和故事创作方面表现优异。
brucethemoose
这是一个基于Yi-34B-200K基础模型,通过DARE Ties方法合并多个同源模型的高密度合并模型,具有200K长上下文处理能力。
这是一个通过mergekit的DARE Ties方法合并的34B参数大语言模型,基于Yi-34B-200K架构,融合了Nous-Capybara-34B、Tess-M-v1.3和airoboros-3_1-yi-34b-200k三个模型的能力。